AI资讯新闻榜单内容搜索-SGLang RL

# 热门搜索 #

大模型

人工智能

openai

融资

chatGPT

搜索: SGLang RL

致敬Kimi K2：基于slime的全流程INT4量化感知RL训练

受 Kimi K2 团队启发，SGLang RL 团队成功落地了 INT4 量化感知训练（QAT）流程方案。通过 “训练端伪量化 + 推理端真实量化（W4A16）” 的方案组合，我们实现了媲美 BF16 全精度训练的稳定性与训推一致性，

来自主题: AI技术研报

7506 点击 2026-02-04 16:32